AI视频提示词怎么写?Seedance 2.0七步公式,从翻车到电影级

2026-07-27 11:47:45 72 AI智能编辑QW Seedance AI创作 AI生成 AI AI视频 AIGC 提示词

Seedance 2.0 七步提示词公式封面

同样是用 Seedance 2.0 生成视频,有人拍出了光影细腻、运镜丝滑的电影级短片,有人却做出了人物变形、画面抽搐的"恐怖谷"素材。工具一样,模型一样,为什么差距这么大?答案只有一个:提示词
Seedance 2.0 是字节跳动出品的 AI 视频生成工具,在即梦平台即可使用,支持文字、图片、音频、视频四种模态输入。它的能力上限很高,但能不能把上限拉满,完全取决于你怎么"指挥"它。今天这篇文章,我们把一套经过大量实测验证的七步提示词公式拆给你看——按这个顺序写,AI 才能看懂你要什么。

核心心法:不是写散文,是写拍摄清单

很多人写提示词像在写抒情散文:"一个孤独的女孩走在雨中,眼神里满是忧伤……"画面感是有了,但 AI 根本不知道该怎么拍。正确的思路是:把提示词当成给 AI 写的导演拍摄清单。每一条信息都要可执行、可量化、可验证。你要告诉它:谁、在哪、做什么、怎么拍、不要什么——像交代摄影师一样交代清楚,而不是让 AI 去"脑补"你的文艺想象。

Seedance 2.0 七步万能公式流程图

一、七步万能公式——按这个顺序写,AI 才能看懂

Seedance 2.0 的信息处理是有优先级的:素材锁定 > 动作拆解 > 一致性约束 > 运镜 > 场景光影 > 画质。我们按照这个优先级,把提示词拆成七步:
1
素材锁定。如果你有参考图片,第一步就是明确告诉 AI 哪些元素不可更改。比如"参考附图中的建筑外观,保持其哥特式尖顶和红色砖墙不变"。这一步是给 AI 画一条红线——哪些东西是"铁打的",不许动。
2
主体定义。用可量化的客观外貌特征描述人物或物体,比如"25岁左右的亚洲女性,黑色齐肩短发,穿白色衬衫和深蓝色牛仔裤"。不要用"美丽""帅气""有气质"这种主观词,AI 理解不了,每次生成结果都不一样。
3
动作拆解。把连续动作按时间轴拆成微动作。比如"0-3秒:右手缓缓抬起;3-7秒:手指轻触窗玻璃;7-10秒:微微转头看向镜头"。10 秒以内的视频,动作不要超过 3 个,否则 AI 会手忙脚乱。
4
场景光影。写明具体的时间、地点、光线方向和色温。比如"傍晚6点,海边栈道,夕阳从人物左后方45度照射,暖橙色光线,色温约3200K"。越具体,AI 越不需要自己"脑补"光影逻辑。
5
运镜指令。只写 1-2 种镜头运动方式,比如"缓慢推进"或"从左向右平移"。千万不要堆砌——"推进+拉远+旋转+环绕"全写上,AI 会直接摆烂,运镜逻辑会崩。
6
一致性约束。强制要求帧间过渡自然、人物不变形。比如"全程保持人物面部特征一致,肢体比例不变,帧间过渡平滑无跳变"。这一步常被忽略,但它恰恰是区分"专业感"和"廉价感"的关键。
7
负面排除。明确列出你不想看到的元素。比如"不要模糊、不要肢体畸形、不要水印、不要文字乱码、不要画面闪烁"。AI 有时会自由发挥加你不想要的东西,负面提示词就是它的边界线。

二、3 组正反案例对比——看完秒懂差距

案例一:人物行走镜头
❌ 错误示范:"一个美女走在街上,很好看,电影感。"
✅ 正确示范

【素材锁定】参考附图人物形象,服装与发型不可更改。

【主体】30岁亚洲男性,短发,穿灰色风衣和黑色长裤,手持黑色公文包。

【动作】0-4秒:右脚迈出,步伐稳健;4-8秒:继续前行,目视前方;8-10秒:微微抬眼看向镜头方向。

【场景】上午10点,上海陆家嘴街道,阳光从右侧照射,色温5500K,路面有轻微反光。

【运镜】镜头缓慢跟拍,保持人物在画面中央。

【约束】全程人物面部一致,肢体比例自然,帧间过渡平滑。

【排除】不要模糊、不要肢体变形、不要水印。

案例二:产品展示镜头
❌ 错误示范:"一个很酷的手机在旋转,背景很炫,8K超高清。"
✅ 正确示范

【素材锁定】参考附图中手机外观,颜色与造型不可更改。

【主体】银色直板智能手机,6.7英寸屏幕,背面三摄模组,金属中框。

【动作】0-5秒:手机绕Y轴匀速旋转180度;5-10秒:继续旋转至360度回到正面。

【场景】纯黑色背景,顶部柔光箱打光,光线从正上方垂直照射,色温6500K。

【运镜】固定机位,镜头不动。

【约束】手机形状全程保持一致,屏幕反光自然,帧间无跳变。

【排除】不要背景杂乱、不要手机变形、不要出现水印或文字。

案例三:带音效的叙事短片
❌ 错误示范:"一个人在咖啡馆里说话,有背景音乐,很有氛围。"
✅ 正确示范

【素材锁定】参考附图中咖啡馆内景和人物形象。

【主体】28岁亚洲女性,扎低马尾,穿米色针织衫,坐在木质桌前。

【动作】0-3秒:低头看手中的咖啡杯;3-6秒:缓缓抬头微笑;6-10秒:开口说话,嘴唇自然开合。

【场景】下午3点,日式咖啡馆内部,窗外自然光从左侧照入,室内暖黄灯光,色温3000K。

【运镜】缓慢推进,从中景推至近景。

【音效】(轻柔爵士钢琴BGM) <咖啡机蒸汽声> {台词:"今天的拿铁,味道不错。"} 【字幕:今天的拿铁,味道不错。】

【约束】人物面部全程一致,口型与台词匹配,帧间过渡平滑。

【排除】不要模糊、不要面部变形、不要环境音过大盖过人声。

音画分离符号体系
案例三里的符号是有讲究的:背景音乐用 ()、环境音效用 <>、台词用 {}、字幕用 【】。这套体系能让 AI 精确区分不同类型的音频元素,不会把台词当成旁白,也不会把环境音当成 BGM。

4个容易踩的坑 避坑对照图

三、4 个容易踩的坑

坑一:描述太模糊。"一个好看的人在一个好看的地方"——这种提示词等于没写。AI 会随机填充所有细节,每次结果都不一样,完全无法控制。解决:所有关键信息都要具体到可量化的程度。
坑二:堆砌画质关键词。"8K超高清、HDR、电影级画质、光线追踪、虚幻引擎5……"写了一堆,但对画面内容没有任何帮助。Seedance 2.0 的画质主要由模型本身决定,堆砌这些词不会让画面更好,反而分散 AI 对内容指令的注意力。
坑三:多种运镜混用。"镜头先推进再拉远然后旋转最后环绕"——AI 在10秒内处理不了这么复杂的运镜序列,结果就是运镜逻辑崩溃,画面抖动或撕裂。解决:一次只用 1-2 种运镜,复杂的镜头运动拆成多段分别生成再剪辑。
坑四:情绪词太抽象。"充满张力的眼神""令人心碎的表情"——AI 不知道"张力"和"心碎"长什么样。它需要的是可执行的描述:"眉头微皱,嘴角下压,目光直视镜头"。把情绪翻译成具体的面部肌肉动作,AI 才能精准还原。

写在最后

AI 视频生成不是"输入一句话,等待奇迹"的魔法,而是一门需要精确表达的"技术活"。Seedance 2.0 的七步公式本质上就是一套结构化沟通协议——你用 AI 能理解的方式告诉它你要什么,它才能给你想要的结果。
这套公式不需要你死记硬背,把它保存下来,每次写提示词的时候对照着检查一遍。写多了,你自然会形成"给 AI 写拍摄清单"的思维习惯。从今天开始,告别翻车视频,用七步公式写出你的第一个电影级镜头。

选择样式

选择布局
选择颜色
选择背景图案
选择背景图片